導讀:Mozilla希望讓初創(chuàng)公司,研究人員和業(yè)余愛好者更容易構建支持語音的應用,服務和設備。為此,它今天發(fā)布了最新版本的Common Voice,這是一個開源的語音數(shù)據(jù)集,現(xiàn)在包括來自42000名貢
發(fā)表日期:2019-09-02
文章編輯:興田科技
瀏覽次數(shù):9983
標簽:
Mozilla希望讓初創(chuàng)公司,研究人員和業(yè)余愛好者更容易構建支持語音的應用,服務和設備。為此,它今天發(fā)布了最新版本的Common Voice,這是一個開源的語音數(shù)據(jù)集,現(xiàn)在包括來自42000名貢獻者超過1400小時的語音樣本,涵蓋18種語言,包括包括英語、法語、德語、荷蘭語、Hakha Chin語、世界語、波斯語、巴斯克語、西班牙語、中文、威爾士語和卡布語。
Mozilla聲稱,它是同類語言中最大的多語言數(shù)據(jù)集之一,比8個月前公開的普通語音語料庫要大得多,其中包含了2萬名英語志愿者500小時,40萬份錄音,而且語料庫很快就會擴大。該組織表示,70種語言的數(shù)據(jù)收集工作正在通過通用語音 網(wǎng)站 和移動應用程序積極開展。
通用語音可以集成到Deepspeech中,這是一套由Mozilla的機器學習小組維護的開源的語音到文本、文本到語音引擎和經(jīng)過培訓的模型,它不僅包含語音片段,還包含一些自愿者提供的元數(shù)據(jù),這些元數(shù)據(jù)可用于培訓語音引擎,如演講者的年齡、性別等等。
為了簡化流程,Mozilla本周推出了一款改進的Common Voice網(wǎng)絡工具,可以根據(jù)不同的提示進行剪輯,還提供了用于查看、重新錄制和跳過剪輯的新控件。此外,它還推出了新的配置文件功能,允許用戶跨語言跟蹤進度和指標,并添加人口統(tǒng)計信息。Mozilla表示,在接下來的幾個月里,它將嘗試不同的方法來通過社區(qū)努力和新的合作伙伴關系,增加數(shù)據(jù)的數(shù)量和質(zhì)量。最終目標旨在為那些尋求構建和使用語音技術的人提供更多更好的語音數(shù)據(jù)。
【來源:cnBeta.COM】
更多新聞
2020
魯沒有武德,公然揭露雷軍的短命,小米在不義,米粉:規(guī)規(guī)矩矩無聊的手機會議也是一樣,有趣的盧脫口秀更是萬里挑一。這一次,魯向羅永浩致敬,把紅米Note 9系列發(fā)布會拍成脫口秀,給名
View details
2020
11月小米新機第一次體驗:一個不發(fā)燒生的驚人耐力怪獸終極性價比是Redmi獨立運營后的產(chǎn)品理念。這一年,概念可以詮釋到極致。從紅米K30到紅米K30S,幾乎每一款手機都是相應檔位
View details
2020
諾貝爾獎獲得者朱的最新演講:如果你不開心,你可能會走錯路!諾獎得主朱棣文:我有一些人生經(jīng)驗,和年輕科學家分享論壇 演講第三屆世界頂尖科學家論壇特設科學態(tài)度大師講堂,由世界
View details
2020
中國手機“挺進”美國市場,三個月內(nèi)售出220萬部,僅次于LG目前,中國手機品牌在全球市場上風頭正勁。即使華為被美國制裁,手機海外銷量大幅下滑,但小米、OPPO、vivo等品牌的強勢
View details